Scaling 的不只是模型:EvoX 想做下一个入口
Scaling 的不只是模型:EvoX 想做下一个入口EvoMap团队推出自进化智能体EvoX,采用无中心调度的蜂群模式让大量Agent平级协作、自主组队,在563道逻辑、数学、物理题上将Claude Haiku 4.5的正确率从单Agent的26.29%提升至70%以上,并开源AutoResearch项目构建Agent经验基础设施。
搜索
EvoMap团队推出自进化智能体EvoX,采用无中心调度的蜂群模式让大量Agent平级协作、自主组队,在563道逻辑、数学、物理题上将Claude Haiku 4.5的正确率从单Agent的26.29%提升至70%以上,并开源AutoResearch项目构建Agent经验基础设施。
Claude Fable 5.1发布数小时内即遭知名黑客Pliny the Liberator越狱,其在GitHub公开泄露了超27万字的完整系统提示词,曝光了模型的安全规则、记忆禁区及46个内置工具架构等核心细节。
一觉醒来,Anthropic再次改写了机器智能的坐标系。
Anthropic 发布 Claude Fable 5.1 和 Claude Mythos 5.1,Fable 5.1 多项基准测试超越上一代,缓存读取成本降低 75%,典型任务整体费用降低约 25%、高 Agent 化任务最高降低约 45%,Mythos 5.1 则面向经审核的高风险领域合作伙伴提供更宽松能力并采用更严格的访问控制。
“你如果不能在几个小时内重建 Cursor,下次面试会非常艰难——那不过是 300 行代码的一个 while 循环。”
GitHub热榜第一的开源项目Archify是一款可嵌入Claude Code等AI编程Agent的架构图生成工具,能将代码仓库一键转化为可搜索、可交互的HTML格式架构图,其开发者"也无风雨也雾晴"凭借该项目从专升本背景成功斩获上海大厂Offer。
OpenClaw数月内GitHub Star飙至38万成现象级爆款,但因Token消耗与安全风险被Claude Code、Codex等Harness取代而迅速降温,国内已涌现30余款衍生产品,创始人Peter Steinberger已加入OpenAI研发下一代Agent。
Ornith-1.5采用模型自出题、自搭脚手架、自跑轨迹的三段式强化学习闭环,在Terminal-Bench 2.1自测中以86.1分超过其自测的Claude Opus 4.8(85.0分),较两个月前的1.0版本提升约11%。
Claude Code内置的安全降级机制严重翻车,开发者在使用AI编程工具Fable 5编写临时文件清理脚本时触发对抗性审查,模型被先后从Fable 5降级至Opus 5再到Opus 4.8,最终因变量复用错误导致Opus 4.8误删开发者Guillemot的整个主目录,700GB数据丢失。
Anthropic正式宣布:Claude Chat和云端Claude Cowork,从今天起共用同一套记忆。Claude记忆从此无处不在,而且,你能决定它记住什么。Claude Code之父Boris Cherny转发了这条公告,称它是一个小改进:记忆现在更简单也更强了。